新世代の具現化推論モデル「Gemini Robotics ER2」が発表。ハードウェア向けに設計され、物理環境の理解と多段階タスク計画能力を大幅に向上。さらに、マルチロボット協調作業の課題を初めて克服し、人型ロボットの実用化を加速する。....
Google DeepMindは新たな音楽生成モデルであるLyria 3.5を発表しました。音楽性、歌詞および人声の表現力、そして制作のコントロールにおいて大幅に向上しており、より複雑で自然なメロディー構造を構築できるようになり、AI音楽がプロフェッショナルな応用へと進展しています。
グーグルDeepMindは、ノーベル化学賞受賞のAlphaFoldチームを解散。中心人物のハサビス氏と江珀氏は2024年に受賞するが、主要論文の著者の多くは既に他プロジェクトへ異動。スター研究者チームが静かに解体されている。....
グーグルDeepMindは従業員の士気低下でGemini 3.5 Proの発表を延期、計画より数か月遅れ。小規模モデルも評価が分かれ、Meta AI責任者に嘲笑される。軍契約が離職を加速させ、チームは人材流出に苦しむ。共同責任者ノーム・シャジールも退社と報じられた。....
Veo 4 は Google DeepMind の AI 動画生成と画像編集プラットフォームです。
Google DeepMindの旗艦的なマルチモーダルAIで、100万トークンのコンテキストを持ち、博士レベルの推論能力と高度なコーディング能力を備えています。
Nano Banana 2 は Google DeepMind が開発したプロフェッショナルな AI 画像編集ツールです。
Google DeepMindが開発した、最先端のAI天気予報技術です。
Google
-
入力トークン/百万
出力トークン/百万
コンテキスト長
$0.14
$0.28
131
$1
$17.5
$70
2.1k
brittlewis12
Gemma 3 4B IT GGUFはGoogle DeepMindが開発した軽量オープンソース言語モデルで、Geminiモデルと同じ研究と技術に基づいて構築されています。このモデルは128Kの大きなコンテキストウィンドウを持ち、140種類以上の言語をサポートし、GGUF形式を採用しているため、さまざまなデバイスでの展開と実行が容易です。
Gemma 3 1B IT GGUFは、Google DeepMindが開発した軽量オープンソース言語モデルのGGUF形式のバージョンです。このモデルは、Gemma 3 1B IT(命令微調整)モデルを基に変換され、128Kの大きなコンテキストウィンドウを持ち、140種類以上の言語をサポートし、リソースが限られた環境でのデプロイに適しています。
Crystalcareai
GemMoEは、Deepmindのジェンマアーキテクチャに基づく専門家混合(MoE)モデルであり、8つの個別に微調整されたジェンマモデルを融合し、各トークンに2人の専門家を備えており、強力でトレーニングと推論が容易です。
HuggingFaceM4
IDEFICSはDeepmindが開発したクローズドソースの視覚言語モデルFlamingoのオープンソース再現版で、マルチモーダル入力(画像+テキスト)をサポートし、テキスト出力を生成します。
IDEFICSはDeepmindが開発したクローズドソースの視覚言語モデルFlamingoのオープンソース再現版で、任意のシーケンスの画像とテキスト入力を受け取り、テキスト出力を生成できるマルチモーダルモデルです。
IDEFICSはオープンソースのマルチモーダルモデルで、画像とテキスト入力を処理しテキスト出力を生成できます。Deepmind Flamingoモデルのオープンソース再現版です。
IDEFICS-9Bは90億パラメータのマルチモーダルモデルで、画像とテキスト入力を処理しテキスト出力を生成できます。DeepmindのFlamingoモデルのオープンソース再現版です。
oandreae
このモデルはdeepmind/language-perceiverをfinancial_phrasebankデータセットでファインチューニングした金融テキスト感情分類モデルです。
deepmind
BERTに基づくマスク言語モデリングタスクで事前学習され、UTF - 8バイト入力をサポートするマルチモーダルTransformerモデル
ImageNetで事前学習された汎用ビジュアルパーサーバーモデルで、学習型位置埋め込みを用いて画像入力を処理します。
ImageNetで事前学習された汎用視覚パーシバーモデルで、畳み込み前処理とトランスフォーマーアーキテクチャを採用し、画像分類タスクをサポート
Perceiver IOは、複数のモーダルデータを処理できる汎用Transformerアーキテクチャです。このモデルは画像分類タスク用に設計され、ImageNetデータセットで事前学習されています。